iT邦幫忙

2026 iThome 鐵人賽

DAY 7
0
AI Security

淺談OWASP Top 10 for Large Language Model Applications系列 第 7

淺談OWASP Top 10 for LLM Applications-Prompt Injection 怎麼防

  • 分享至 

  • xImage
  •  

Day 7|Prompt Injection 怎麼防?

前兩篇介紹了 Prompt Injection 的概念與常見攻擊場景,最後一篇就來看看:面對 Prompt Injection,我們可以怎麼防?

Prompt Injection 很難單純靠一條規則完全阻擋,因此通常需要從多個層面一起防禦。

  1. 限制 LLM 的權限

不要讓 LLM 擁有不必要的權限。

例如 AI 只是負責回答問題,就不需要讓它直接修改資料庫或執行重要系統操作。

  1. 區分指令與資料

要盡量讓 Application 能夠區分:

「這是系統真正的指令」

「這只是使用者或外部資料提供的內容」

尤其在 RAG、文件分析等情境下,不能把所有內容都當成可信任的指令。

  1. 驗證模型輸出

LLM 產生的內容不應該直接被當成可信任的結果。

如果模型的輸出會進一步執行 SQL、呼叫 API 或操作其他系統,就應該經過適當的驗證與限制。

  1. 高風險操作加入人工確認

對於刪除資料、付款、寄送重要 Email 等高風險操作,可以要求使用者再次確認,而不是讓 AI 自己決定並直接執行。

可以看到,Prompt Injection 的防禦重點並不是「想辦法讓 AI 永遠不被騙」,而是:

即使 LLM 被成功誘導,也不要讓一次錯誤的輸出直接造成嚴重的安全影響。

這其實也是 LLM Application Security 很重要的思維:不要只相信模型,要在模型之外建立安全控制。


上一篇
淺談OWASP Top 10 for LLM Applications-Prompt Injection 的攻擊場景
下一篇
淺談OWASP Top 10 for LLM Applications-Sensitive Information Disclosure 是什麼
系列文
淺談OWASP Top 10 for Large Language Model Applications10
圖片
  熱門推薦
圖片
{{ item.channelVendor }} | {{ item.webinarstarted }} |
{{ formatDate(item.duration) }}
直播中

尚未有邦友留言

立即登入留言